英伟达
2026-08-25 12:37:13英伟达称 Groq 3 LPX 已全面投产,Gemma 4 31B 推理达 3400 token/秒
英伟达宣布 Groq 3 LPX 推理芯片已进入全面生产阶段,并称其在 Gemma 4 31B 模型上的推理速度达到每秒 3400 token。按英伟达说法,这一速度比 Cerebras 快 4 倍。不过报道同时提到,这一对比并不简单:英伟达至少需要 64 个加速器才能达到该速度,而 Cerebras 仅需 1 至 2 个。该架构在大型 MoE 模型上的扩展能力仍有待观察。
10



